即時快訊
AI助零售商精準預測假期商品組合 轉向「狹而深」策略 全球市場波動加劇 新加坡年輕投資者轉向本地股市尋求避險 美國數據中心爭議升溫 「中國介入」說法與地方居民反彈交鋒 矽谷IEM擲2億美元於聖安東尼奧設廠 助德州製造業增三千工作 三菱日聯銀行捨棄效率至上思維 轉向客戶生命週期價值經營 支付鏈趨複雜 金融監管挑戰「見林不見樹」防洗錢 Label Studio 助甲骨文雲 AI 視覺服務 客製模型訓練更高效 英國改革黨擬推十年來最大規模監管鬆綁 減稅助中小企擺脫歐盟法規 房地產迎AI新時代 Roomvu、Lofty推工具助房仲提升搜尋能見度 韓國新創平台與全球資料庫聯手 助當地企業擴展國際能見度
圖/本報資料庫
AI模型
a few seconds ago

#AI模型
#大型語言模型
#邊緣運算
#Multiverse Computing
#OpenAI
圖/本報資料庫
圖/本報資料庫
商傳媒|林昭衡/綜合外電報導
摘要

Multiverse Computing 研究團隊發表了一種名為「Quantization-Aware Healing」的新方法,成功將 OpenAI 的大型語言模型 GPT-OSS 縮小一半參數並壓縮記憶體,但效能卻超越了原始模型,這項突破性技術有望讓 AI 在低功耗設備上更廣泛地應用。

根據《Decrypt》報導,人工智慧(AI)領域近日出現一項突破性進展。位於美國的 AI 公司 Multiverse Computing 研究團隊於 8 月 25 日在 Hugging Face 部落格上發表了一種名為「Quantization-Aware Healing」的新方法,成功將 OpenAI 開源的 GPT-OSS 大型語言模型(LLM)從 1,200 億個參數(parameters)縮小至 600 億個,同時將模型記憶體壓縮至 4 位元,但效能卻不減反增。

一般而言,AI 模型參數越多、記憶體需求越大,效能通常也越強。但這項新技術顛覆了傳統認知,經測試發現,這款縮小後的 GPT-OSS 模型在九項評估測試中,有七項超越了原始的全參數模型。研究人員解釋,「Quantization-Aware Healing」方法並非簡單地壓縮,而是讓縮小的模型回頭向未壓縮的原始模型學習,確保在壓縮過程中能「修復」因資料量減少可能造成的智慧損失。

此技術的實用價值在於,量化(Quantization)步驟不再僅是降低成本的手段,更成為提升模型品質的機會。透過這種方式,模型在經過「治療」後,所需的記憶體約為原始模型的四分之一,參數數量減半,卻能提供同等或更高的準確度。這意味著 AI 模型未來可在更便宜、記憶體更小的邊緣運算設備上運行,大幅降低服務成本並擴大應用範圍。

Multiverse Computing 已將這款經過改良、名為 Hypernova-60B 的模型以開放權重(open weights)的形式釋出在 Hugging Face 平台上。